隨著 LLM 快速發展,身為剛入行不久的junior,深刻體會到AI專案開發迭代的速度。
回顧這幾年,從2022年各自摸索模型訓練、進展到基於成熟開源模型的微調(Fine-tuning),再到如今全面聚焦於系統工作流(Workflow) 的編排。
原先想單純以「Agent」為題,但實務上,能讓Agent穩定發揮價值的關鍵,往往在於背後工作流與工程管線的設計。
在接下來的28+1天裡,我會依序介紹現代Agent工程的核心技術、如何將它們落地於實際工作流,以及各自適合的應用場景。希望透過這趟挑戰,梳理完整的技術拼圖,也提升自己在架構規劃上的認知與視野!
| 天數 | 文章標題 | 核心主軸與重點 |
|---|---|---|
| Day 2 | 【Day 2】甚麼是 Prompt Engineering | CoT、Few-shot、Role Prompting 與邊界約束 |
| Day 3 | 【Day 3】怎麼應用 Prompt Engineering | 工作流中的動態提示詞模組化與模板管理 |
| Day 4 | 【Day 4】甚麼是 Context Engineering | 上下文視窗管理、Token 預算與關聯度排序 |
| Day 5 | 【Day 5】怎麼應用 Context Engineering | 打造高效 Context 壓縮、過濾與長文本注入流 |
| Day 6 | 【Day 6】甚麼是 Structured Output Engineering | JSON Schema、Pydantic、Type-safe 輸出保證 |
| Day 7 | 【Day 7】怎麼應用 Structured Output Engineering | 將 LLM 輸出無縫銜接下游 API 與關聯式資料庫 |
| Day 8 | 【Day 8】甚麼是 Tool Calling Engineering | Function Calling 運作原理與工具描述定義 |
| Day 9 | 【Day 9】怎麼應用 Tool Calling Engineering | 多工具鏈路調用、參數容錯與動態工具選擇 |
| Day 10 | 【Day 10】甚麼是 Retrieval Engineering (RAG) | 語義檢索、向量切分與 Hybrid Search 架構 |
| Day 11 | 【Day 11】怎麼應用 Retrieval Engineering | 整合 RAG 工作流:Rerank、動態 Chunking 實戰 |
| Day 12 | 【Day 12】甚麼是 Memory Engineering | 短期會話緩存、長期語意記憶與外部儲存機制 |
| Day 13 | 【Day 13】怎麼應用 Memory Engineering | 跨對話上下文摘要、記憶提取與用戶畫像沉澱 |
| Day 14 | 【Day 14】甚麼是 Routing & Workflow Engineering | 意圖識別、條件分支與線性/圖形工作流引擎 |
| Day 15 | 【Day 15】怎麼應用 Routing & Workflow Engineering | 用狀態機(State Machine)實現複雜業務邏輯分流 |
| Day 16 | 【Day 16】甚麼是 Multi-Agent Engineering | 多智能體角色分工、通訊協議與協同拓撲 |
| Day 17 | 【Day 17】怎麼應用 Multi-Agent Engineering | 實作「規劃者-執行者-審查者」協作工作流 |
| Day 18 | 【Day 18】甚麼是 Human-in-the-Loop (HITL) | 人機協作邊界、關鍵節點審批與例外中斷機制 |
| Day 19 | 【Day 19】怎麼應用 Human-in-the-Loop | 在敏感流程中加入人工覆核、即時干預與回饋循環 |
| Day 20 | 【Day 20】甚麼是 Harness Engineering | 測試沙盒、環境隔絕、模擬工具與執行保護 |
| Day 21 | 【Day 21】怎麼應用 Harness Engineering | 打造安全的 Agent 代碼執行環境與自動化測試套件 |
| Day 22 | 【Day 22】甚麼是 Guardrails & Safety Engineering | 提示注入防禦、輸出安全過濾與幻覺校驗 |
| Day 23 | 【Day 23】怎麼應用 Guardrails & Safety Engineering | 部署前置/後置驗證管道(Validation Pipeline) |
| Day 24 | 【Day 24】甚麼是 Evaluation Engineering (Evals) | LLM-as-a-Judge、基準測試集構建與指標設計 |
| Day 25 | 【Day 25】怎麼應用 Evaluation Engineering | 建立自動化 CI/CD 工作流的 Agent 評測體系 |
| Day 26 | 【Day 26】甚麼是 Observability & Tracing | Token 追蹤、鏈路調試(Traces)與延遲監控 |
| Day 27 | 【Day 27】怎麼應用 Observability & Tracing | 整合 LangSmith / Phoenix 進行排錯與成本分析 |
| Day 28 | 【Day 28】甚麼是 AgentOps | 從開發到生產環境的部署、版本控制與回滾機制 |
| Day 29 | 【Day 29】怎麼應用 AgentOps | 建構高可用、低延遲的企業級 Agent 線上維運流 |
| Day 30 | 【Day 30】30天全景彙整:從零件到系統,建構現代 Agent 工程心法 | 總結 30 天模組,串聯完整工程落地體系與未來展望 |